Thyroid Cancer Risk Prediction from Multimodal Datasets Using Large Language Model
Die Studie stellt ein multimodales Deep-Learning-Framework vor, das mittels Vision Transformer und einem sprachbasierten Modell MRT-Bilder mit klinischen Textdaten kombiniert, um die Genauigkeit der präoperativen Vorhersage von Schilddrüsenkrebs im Vergleich zu unimodalen Ansätzen signifikant zu verbessern.